"language model" meaning in All languages combined

See language model on Wiktionary

Noun [English]

Forms: language models [plural]
Head templates: {{en-noun}} language model (plural language models)
  1. (machine learning) A machine learning model that assigns probabilities to sequences of characters or words, and/or is capable of generating plausible subsequent text from a given prompt. Wikidata QID: Q3621696 Synonyms: LM Hypernyms: model Derived forms: large language model, small language model Translations (ML model): լեզվի մոդել (english: lezvi model) (Armenian), моўная мадэль (mównaja madelʹ) [feminine] (Belarusian), taalmodel [neuter] (Dutch), kielimalli (Finnish), ენობრივი მოდელი (enobrivi modeli) (Georgian), Sprachmodell [neuter] (German), modelo de linguagem [masculine] (Portuguese), model de limbă [neuter] (Romanian), языкова́я моде́ль (jazykovája modélʹ) [feminine] (Russian), språkmodell [common-gender] (Swedish), мовна модель (movna modelʹ) [feminine] (Ukrainian)

Inflected forms

Alternative forms

{
  "forms": [
    {
      "form": "language models",
      "tags": [
        "plural"
      ]
    }
  ],
  "head_templates": [
    {
      "args": {},
      "expansion": "language model (plural language models)",
      "name": "en-noun"
    }
  ],
  "lang": "English",
  "lang_code": "en",
  "pos": "noun",
  "senses": [
    {
      "categories": [
        {
          "kind": "other",
          "name": "English entries with incorrect language header",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Entries with translation boxes",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Pages with 1 entry",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Pages with entries",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Terms with Armenian translations",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Terms with Belarusian translations",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Terms with Dutch translations",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Terms with Finnish translations",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Terms with Georgian translations",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Terms with German translations",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Terms with Portuguese translations",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Terms with Romanian translations",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Terms with Russian translations",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Terms with Swedish translations",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "name": "Terms with Ukrainian translations",
          "parents": [],
          "source": "w"
        },
        {
          "kind": "other",
          "langcode": "en",
          "name": "Machine learning",
          "orig": "en:Machine learning",
          "parents": [],
          "source": "w"
        }
      ],
      "derived": [
        {
          "word": "large language model"
        },
        {
          "word": "small language model"
        }
      ],
      "examples": [
        {
          "bold_text_offsets": [
            [
              17,
              32
            ]
          ],
          "ref": "2022 [2009], Chengxiang Zhai, Statistical Language Models for Information Retrieval, Springer Nature, →ISBN, page 9:",
          "text": "Although unigram language models are simple, they clearly make unrealistic assumptions about word occurrences in text.",
          "type": "quotation"
        }
      ],
      "glosses": [
        "A machine learning model that assigns probabilities to sequences of characters or words, and/or is capable of generating plausible subsequent text from a given prompt."
      ],
      "hypernyms": [
        {
          "word": "model"
        }
      ],
      "id": "en-language_model-en-noun-en:Q3621696",
      "links": [
        [
          "machine learning",
          "machine learning"
        ],
        [
          "machine learning",
          "machine learning"
        ],
        [
          "model",
          "model"
        ],
        [
          "probabilities",
          "probability"
        ],
        [
          "sequences",
          "sequences"
        ],
        [
          "character",
          "character"
        ],
        [
          "word",
          "word"
        ],
        [
          "generating",
          "generate"
        ],
        [
          "plausible",
          "plausible"
        ],
        [
          "text",
          "text"
        ],
        [
          "prompt",
          "prompt"
        ]
      ],
      "qualifier": "machine learning",
      "raw_glosses": [
        "(machine learning) A machine learning model that assigns probabilities to sequences of characters or words, and/or is capable of generating plausible subsequent text from a given prompt."
      ],
      "senseid": [
        "en:Q3621696"
      ],
      "synonyms": [
        {
          "word": "LM"
        }
      ],
      "translations": [
        {
          "code": "hy",
          "english": "lezvi model",
          "lang": "Armenian",
          "lang_code": "hy",
          "sense": "ML model",
          "translation": "lezvi model",
          "word": "լեզվի մոդել"
        },
        {
          "code": "be",
          "lang": "Belarusian",
          "lang_code": "be",
          "roman": "mównaja madelʹ",
          "sense": "ML model",
          "tags": [
            "feminine"
          ],
          "word": "моўная мадэль"
        },
        {
          "code": "nl",
          "lang": "Dutch",
          "lang_code": "nl",
          "sense": "ML model",
          "tags": [
            "neuter"
          ],
          "word": "taalmodel"
        },
        {
          "code": "fi",
          "lang": "Finnish",
          "lang_code": "fi",
          "sense": "ML model",
          "word": "kielimalli"
        },
        {
          "code": "ka",
          "lang": "Georgian",
          "lang_code": "ka",
          "roman": "enobrivi modeli",
          "sense": "ML model",
          "word": "ენობრივი მოდელი"
        },
        {
          "code": "de",
          "lang": "German",
          "lang_code": "de",
          "sense": "ML model",
          "tags": [
            "neuter"
          ],
          "word": "Sprachmodell"
        },
        {
          "code": "pt",
          "lang": "Portuguese",
          "lang_code": "pt",
          "sense": "ML model",
          "tags": [
            "masculine"
          ],
          "word": "modelo de linguagem"
        },
        {
          "code": "ro",
          "lang": "Romanian",
          "lang_code": "ro",
          "sense": "ML model",
          "tags": [
            "neuter"
          ],
          "word": "model de limbă"
        },
        {
          "code": "ru",
          "lang": "Russian",
          "lang_code": "ru",
          "roman": "jazykovája modélʹ",
          "sense": "ML model",
          "tags": [
            "feminine"
          ],
          "word": "языкова́я моде́ль"
        },
        {
          "code": "sv",
          "lang": "Swedish",
          "lang_code": "sv",
          "sense": "ML model",
          "tags": [
            "common-gender"
          ],
          "word": "språkmodell"
        },
        {
          "code": "uk",
          "lang": "Ukrainian",
          "lang_code": "uk",
          "roman": "movna modelʹ",
          "sense": "ML model",
          "tags": [
            "feminine"
          ],
          "word": "мовна модель"
        }
      ],
      "wikidata": [
        "Q3621696"
      ]
    }
  ],
  "word": "language model"
}
{
  "derived": [
    {
      "word": "large language model"
    },
    {
      "word": "small language model"
    }
  ],
  "forms": [
    {
      "form": "language models",
      "tags": [
        "plural"
      ]
    }
  ],
  "head_templates": [
    {
      "args": {},
      "expansion": "language model (plural language models)",
      "name": "en-noun"
    }
  ],
  "lang": "English",
  "lang_code": "en",
  "pos": "noun",
  "senses": [
    {
      "categories": [
        "English countable nouns",
        "English entries with incorrect language header",
        "English lemmas",
        "English multiword terms",
        "English nouns",
        "English terms with quotations",
        "Entries with translation boxes",
        "Pages with 1 entry",
        "Pages with entries",
        "Terms with Armenian translations",
        "Terms with Belarusian translations",
        "Terms with Dutch translations",
        "Terms with Finnish translations",
        "Terms with Georgian translations",
        "Terms with German translations",
        "Terms with Portuguese translations",
        "Terms with Romanian translations",
        "Terms with Russian translations",
        "Terms with Swedish translations",
        "Terms with Ukrainian translations",
        "en:Machine learning"
      ],
      "examples": [
        {
          "bold_text_offsets": [
            [
              17,
              32
            ]
          ],
          "ref": "2022 [2009], Chengxiang Zhai, Statistical Language Models for Information Retrieval, Springer Nature, →ISBN, page 9:",
          "text": "Although unigram language models are simple, they clearly make unrealistic assumptions about word occurrences in text.",
          "type": "quotation"
        }
      ],
      "glosses": [
        "A machine learning model that assigns probabilities to sequences of characters or words, and/or is capable of generating plausible subsequent text from a given prompt."
      ],
      "hypernyms": [
        {
          "word": "model"
        }
      ],
      "links": [
        [
          "machine learning",
          "machine learning"
        ],
        [
          "machine learning",
          "machine learning"
        ],
        [
          "model",
          "model"
        ],
        [
          "probabilities",
          "probability"
        ],
        [
          "sequences",
          "sequences"
        ],
        [
          "character",
          "character"
        ],
        [
          "word",
          "word"
        ],
        [
          "generating",
          "generate"
        ],
        [
          "plausible",
          "plausible"
        ],
        [
          "text",
          "text"
        ],
        [
          "prompt",
          "prompt"
        ]
      ],
      "qualifier": "machine learning",
      "raw_glosses": [
        "(machine learning) A machine learning model that assigns probabilities to sequences of characters or words, and/or is capable of generating plausible subsequent text from a given prompt."
      ],
      "senseid": [
        "en:Q3621696"
      ],
      "synonyms": [
        {
          "word": "LM"
        }
      ],
      "wikidata": [
        "Q3621696"
      ]
    }
  ],
  "translations": [
    {
      "code": "hy",
      "english": "lezvi model",
      "lang": "Armenian",
      "lang_code": "hy",
      "sense": "ML model",
      "translation": "lezvi model",
      "word": "լեզվի մոդել"
    },
    {
      "code": "be",
      "lang": "Belarusian",
      "lang_code": "be",
      "roman": "mównaja madelʹ",
      "sense": "ML model",
      "tags": [
        "feminine"
      ],
      "word": "моўная мадэль"
    },
    {
      "code": "nl",
      "lang": "Dutch",
      "lang_code": "nl",
      "sense": "ML model",
      "tags": [
        "neuter"
      ],
      "word": "taalmodel"
    },
    {
      "code": "fi",
      "lang": "Finnish",
      "lang_code": "fi",
      "sense": "ML model",
      "word": "kielimalli"
    },
    {
      "code": "ka",
      "lang": "Georgian",
      "lang_code": "ka",
      "roman": "enobrivi modeli",
      "sense": "ML model",
      "word": "ენობრივი მოდელი"
    },
    {
      "code": "de",
      "lang": "German",
      "lang_code": "de",
      "sense": "ML model",
      "tags": [
        "neuter"
      ],
      "word": "Sprachmodell"
    },
    {
      "code": "pt",
      "lang": "Portuguese",
      "lang_code": "pt",
      "sense": "ML model",
      "tags": [
        "masculine"
      ],
      "word": "modelo de linguagem"
    },
    {
      "code": "ro",
      "lang": "Romanian",
      "lang_code": "ro",
      "sense": "ML model",
      "tags": [
        "neuter"
      ],
      "word": "model de limbă"
    },
    {
      "code": "ru",
      "lang": "Russian",
      "lang_code": "ru",
      "roman": "jazykovája modélʹ",
      "sense": "ML model",
      "tags": [
        "feminine"
      ],
      "word": "языкова́я моде́ль"
    },
    {
      "code": "sv",
      "lang": "Swedish",
      "lang_code": "sv",
      "sense": "ML model",
      "tags": [
        "common-gender"
      ],
      "word": "språkmodell"
    },
    {
      "code": "uk",
      "lang": "Ukrainian",
      "lang_code": "uk",
      "roman": "movna modelʹ",
      "sense": "ML model",
      "tags": [
        "feminine"
      ],
      "word": "мовна модель"
    }
  ],
  "word": "language model"
}

Download raw JSONL data for language model meaning in All languages combined (3.7kB)


This page is a part of the kaikki.org machine-readable All languages combined dictionary. This dictionary is based on structured data extracted on 2026-09-06 from the enwiktionary dump dated 2026-09-02 using wiktextract (ccec6f1 and 4deed51). The data shown on this site has been post-processed and various details (e.g., extra categories) removed, some information disambiguated, and additional data merged from other sources. See the raw data download page for the unprocessed wiktextract data.

If you use this data in academic research, please cite Tatu Ylonen: Wiktextract: Wiktionary as Machine-Readable Structured Data, Proceedings of the 13th Conference on Language Resources and Evaluation (LREC), pp. 1317-1325, Marseille, 20-25 June 2022. Linking to the relevant page(s) under https://kaikki.org would also be greatly appreciated.